Atac cibernetic fără precedent. Un model de testare OpenAI a evadat și a pătruns în serverele unei companii reale

Scenariul după care funcționează sistemul este cel de „atacator agent”, despre care industria inteligenței artificiale și a securității cibernetice a avertizat că se va întâmpla.

Atac cibernetic fără precedent. Un model de testare OpenAI a evadat și a pătruns în serverele unei companii reale

Scenariul după care funcționează sistemul este cel de „atacator agent”, despre care industria inteligenței artificiale și a securității cibernetice a avertizat că se va întâmpla.

Producătorul ChatGPT a declarat că agentul său - un sistem de inteligență artificială care poate funcționa singur după instrucțiuni umane - a fost testat într-un mediu controlat, dar, după ce a găsit puncte slabe, a reușit să depășească limitele testului.

Este pentru prima oară când un sistem de inteligență artificială își încalcă autonom mediul de testare și ajunge la un sistem extern real, transmit BBC și CNN.

Ca un virus modificat genetic

Scenariul după care funcționează sistemul este cel de „atacator agent”, despre care industria inteligenței artificiale și a securității cibernetice a avertizat că se va întâmpla.

Întregul sistem funcționează ca un virus modificat genetic care scapă dintr-un laborator de bioizolare și apare în sistemele unei instalații vecine.

„Considerăm că acest incident este un incident cibernetic fără precedent, care implică capabilități cibernetice de ultimă generație, și reacționăm în consecință”, a declarat OpenAI într-un comunicat.

„Împărtășim constatările preliminare în această etapă pentru a ajuta să se înțeleagă ce s-a întâmplat și pentru a ajuta la calibrarea a ceea ce modelele sunt acum capabile să facă”, spune compania.

Producătorul ChatGPT a declarat că breșa de securitate a avut loc în timp ce testa intern cât de bune sunt unele dintre noile sale modele la hacking. Modelele se aflau într-un mediu de testare izolat, cunoscut sub numele de sandbox, astfel încât restricțiile normale de siguranță să poată fi dezactivate.

A spart serverele de producție ale Hugging Face și a „rezolvat” exercițiul

Însă OpenAI a declarat că agenții AI au ieșit din sandbox folosind o eroare de securitate necunoscută anterior și au pătruns în sistemele interne ale OpenAI până când au reușit să obțină acces la internet, lucru pe care nu ar fi trebuit să-l aibă.

Odată ce a ajuns online, modelul a considerat că Hugging Face – o companie bine-cunoscută care găzduiește mii de modele și seturi de date de inteligență artificială open-source – avea răspunsul la testul OpenAI. Apoi a spart serverele de producție ale Hugging Face și a extras informațiile necesare pentru a rezolva exercițiul.

Hugging Face observase încălcarea înainte de a ști că era un test OpenAI și a anunțat săptămâna trecută că a detectat o intruziune a unui sistem autonom de agent AI, apoi a raportat incidentul către forțele de ordine. Echipa de securitate a OpenAI a observat separat activitatea neobișnuită pe plan intern, iar cele două companii s-au conectat. Ambele companii spun acum că lucrează împreună pentru a rezolva vulnerabilitățile de securitate exploatate de model.

Citește și:

Orientarea politică a softurilor AI. În ce ideologie crede popularul ChatGPT

„Dr. Apocalipsă”, economistul care a anticipat criza din 2008, avertizează: AI ar putea schimba regula după care au trăit generații întregi. Ce se întâmplă cu joburile și pensiile

 

Distribuie articolul pe:

Lasă un răspuns

Adresa ta de email nu va fi publicată. Câmpurile obligatorii sunt marcate cu *

Ziarul Cotidianul își propune să găzduiască informații și puncte de vedere diverse și contradictorii. Publicația roagă cititorii să evite atacurile la persoană, vulgaritățile, atitudinile extremiste, antisemite, rasiste sau discriminatorii. De asemenea, invită cititorii să comenteze subiectele articolelor sau să se exprime doar pe seama aspectelor importante din viața lor si a societății, folosind un limbaj îngrijit, într-un spațiu de o dimensiune rezonabilă. Am fi de-a dreptul bucuroși ca unii comentatori să semneze cu numele lor sau cu pseudonime decente. Pentru acuratețea spațiului afectat, redacția va modera comentariile, renunțînd la cele pe care le consideră nepotrivite.